AI资讯新闻榜单内容搜索-DeepSeek

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: DeepSeek
曝DeepSeek来了位90后CFO

曝DeepSeek来了位90后CFO

曝DeepSeek来了位90后CFO

DeepSeek据悉将迎来高瓴创投90后合伙人严文韬出任CFO,同时已聘请中信证券筹备上海科创板IPO,并近期发布了DeepSeek V4.1 Flash模型,资本与产品双线加速推进。

来自主题: AI资讯
8530 点击    2026-09-14 18:16
DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash用了哪些黑科技?竟让Flash(差点)逼退Pro

DeepSeek V4.1 Flash技术报告揭秘其通过CED架构对半削减prefill计算、CSA2同时吃满条目/序列/层三个压缩维度、FP4量化main KV缓存及SWA Bounded Replay部署优化等手段,将全局KV缓存压至V4-Flash的1/4、持久化KV压至约1/8,以552B参数实现超越1.6T参数V4 Pro的性能。

来自主题: AI资讯
7878 点击    2026-09-12 19:26
DeepSeek V4.1 Flash 开源:全新架构

DeepSeek V4.1 Flash 开源:全新架构

DeepSeek V4.1 Flash 开源:全新架构

刚刚,DeepSeek 开源了 V4.1 Flash,原生支持视觉理解,也是全新架构系列中最小的一款模型,550B 总参数,输入时激活 8B,输出时激活 16B(你没看错,输入输出激活不同)

来自主题: AI技术研报
7071 点击    2026-09-10 16:58
刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

DeepSeek V4.1 Flash 正式在网页、App 和 API 端全面上线,采用 552B 参数的 MoE 架构与 Causal-Encoder-Decoder 设计,性能全面超越 V4 Pro 并原生支持多模态,DeepSeek Harness v0.1.5 也同步适配。

来自主题: AI资讯
9740 点击    2026-09-10 14:42
独家|DeepSeek今年将扩招到1000人

独家|DeepSeek今年将扩招到1000人

独家|DeepSeek今年将扩招到1000人

9月8日,DeepSeek Harness团队负责人崔添翼在社交平台放出约150个招聘名额,岗位涉及大模型研究平台方向、Agent框架组件方向、研发效率基建方向、数据工程方向等工程师。

来自主题: AI资讯
6871 点击    2026-09-09 11:26
梁文锋听劝,DeepSeek把价格降回来了

梁文锋听劝,DeepSeek把价格降回来了

梁文锋听劝,DeepSeek把价格降回来了

DeepSeek Flash系列自明日中午起降价,闲时缓存、输入和输出价格分别降至每百万Token 0.02元、1元和4元,新模型DeepSeek v4.1 Flash也已上线。

来自主题: AI资讯
8161 点击    2026-09-09 10:30
刚刚,DeepSeek 新模型突然上线,Flash 的模型,Pro 的野心

刚刚,DeepSeek 新模型突然上线,Flash 的模型,Pro 的野心

刚刚,DeepSeek 新模型突然上线,Flash 的模型,Pro 的野心

DeepSeek 突然上线限时内测模型 DeepSeek V4.1 Flash,采用新模型结构并原生支持多模态,在生成速度、使用成本和中文长文写作等实测中表现优于以往版本,DeepSeek 期望其在保持 Flash 速度与价格优势的同时,能力向 V4 Pro 靠拢。

来自主题: AI资讯
10015 点击    2026-09-08 18:06
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。

来自主题: AI技术研报
10122 点击    2026-09-02 09:27